
先说结果
用 WorkBuddy 做短视频,30分钟出一条60秒自媒体成片,不是噱头,是可复制的工作流。核心是"先图后视频"铁律:先用图片快速验证构图和风格(5-10积分/张),满意后再生成视频(50-100积分/条),避免画面翻车浪费积分。本文拆解完整工作流、Prompt五要素公式、视频特效模块和实战案例。
一、WorkBuddy 视频制作三层能力
很多人以为 WorkBuddy 只是"聊天AI",其实在视频这块,它有三层硬实力:
1文生视频:对话里描述画面,生成5-10秒MP4。适合凭空生成动画/创意短片。
2图生视频:给一张图+描述,生成5-10秒MP4。适合让已有画面动起来。
3视频特效:传图+选模板,生成动态特效视频。60+爆款模板,拥抱、变身、万物归尘等。
隐藏技巧
WorkBuddy 内置 ImageGen 图片生成(5-10积分/张),先出图再出视频,是当下最省、最稳的组合拳。图片生成速度快(十几秒出一张),可以快速迭代画面效果,满意后再用这张图生成视频。
怎么触发
打开 WorkBuddy 客户端,在对话框里直接描述你想要的视频画面即可。不需要切换任何模式,WorkBuddy 会自动识别你的意图并调用视频生成能力。
生成一个短视频:一个女孩在落地窗前光脚转圈跳舞,窗外是湖和环山,阳光洒进来,慢动作,电影感
WorkBuddy 会调用文生视频能力,大约2-5分钟后,生成一段5-10秒的短视频,自动保存为MP4格式到你的工作区。
读取 D:\XXX素材 文件夹中的图片和音频,制作 60 秒 16:9 横屏视频,清新风格,自动字幕+轻柔背景音乐,成片保存到桌面
关键点:指令越具体,成片质量越高。只说"做一条职场视频",产出内容会很空洞。标注风格、时长、重点内容,效果会好很多。
二、核心工作流:为什么"先图后视频"是铁律?
视频生成耗积分是图片的 10-20倍(约50-100分/条)。直接文生视频,一旦画面翻车,积分直接打水漂。
正确姿势:三步走
1用图片生成快速验证:构图、人物、风格,十几秒出图,便宜(5-10积分/张),可以快速迭代。
帮我画一张图:一个年轻女行政人员,戴眼镜,穿白衬衫,坐在办公桌前翻阅账本,表情专注,写实风格,柔光,8k超高清
2满意后,拿这张图做图生视频:以图片为基础生成动态视频,人物动作、表情、环境光影都会在原图基础上产生合理的动态变化。
用刚才生成的图片,生成一个短视频:财务人员在办公桌前翻阅账本,表情专注,写实风格,竖屏
3系列视频?固定角色描述关键词:每次生图时,都在Prompt开头加上相同的人物描述,如"年轻女行政人员,戴眼镜,白衬衫,严肃但可靠" + 场景描述。这样不管换什么场景,人物外貌特征都能保持基本一致。
三、Prompt 五要素公式
视频质量80%看提示词。提炼为万能公式:
好Prompt = 镜头角度 + 动作细节 + 环境描写 + 节奏质感 + 否定描述
指令越具体,成片越稳定。
要素1:镜头
镜头角度决定了画面的构图,是视频质量的基础。
常用镜头描述词:全身镜头、半身镜头、特写、俯拍、仰拍、侧面镜头、正面镜头。
要素2:动作
AI需要具体的动作描述才能生成自然的动态画面。写动作时,想象你在给一个没看过这支舞的人描述——他需要知道手怎么动、脚怎么迈、身体怎么转。
比如:"俏皮地转圈跳跃,像蝴蝶一样轻盈"比"跳舞"更生动。
要素3:环境
环境不仅决定了背景,还影响光影效果和整体调性。写环境时,包含三个要素:
如:"窗外是湖和环山,阳光洒进来"能增强画面氛围。
要素4:质感
加入"慢动作""电影感""纪录片风格"等关键词,可以让视频更有质感。这些词会影响AI对镜头运动速度和画面风格的判断。
常用质感词:慢动作、电影感、纪录片风格、清新自然、赛博朋克、复古胶片。
要素5:排雷(否定描述)
AI生成视频和图片时,最常见的Bug是多出肢体、面部异常。在Prompt结尾加上否定描述,可以大幅降低出错率:
only TWO hands visible —— 限定手部数量
anatomically correct hands —— 要求解剖学正确
no extra limbs —— 禁止多余肢体
四、最易出爆款:视频特效模块
视频特效是 WorkBuddy 视频制作中最有趣、最容易出爆款的能力。原理是:你上传一张(或两张)图片,选择一个特效模板,AI会根据模板自动生成一段动态视频。目前支持60+个模板。
热门模板一览
1人物互动:拥抱 hug、亲吻 kissing、比心 hearting、公主抱 bridalcarry
2变装变身:变身机甲 futuresoldier、变身美人鱼 mermaidme、毕业啦 graduation
3物理特效:万物归尘 return2dust、飞走了 balloonfly
4风格转换:动漫视频 animelive、卡通视频 cartoonlive、3D手办风 3dfigure
使用示例
帮我对这张照片应用"万物归尘"特效,让人物化作粒子消散
帮我把这两张单人照片,用"拥抱"模板生成一个相互拥抱的视频
爆款思路
视频特效特别适合做"变装""变身"类短视频内容,传一张人像照,10秒出片。
变装类:赛博朋克、美人鱼、埃及风
互动类:拥抱、亲吻、比心
物理类:万物归尘、气球飞走
爆款逻辑:一张图 + 一个模板 = 零剪辑基础的创意视频。
五、省积分的5条军规
1先图后视频(最重要):先用图片快速迭代,满意后再生成视频。
2调Prompt用低质量参数:调试阶段不用开"8k",正式出片再开高质量。
3固定模板批量产出:不改基准设定,用同一套模板批量生成系列视频。
4不满意先改词再"再来一张":先调整Prompt,而不是直接重新生成。
5每天把积分花在关键画面:免费版额度有限,只对最关键的1-2个画面生成视频,其他用静态图配字幕。
六、实战:30分钟做一条60秒科普口播
主题:为什么早起并不适合所有人。传统流程约4.5小时 → AI流约30分钟,效率近10倍。
0-3分钟:写脚本
让 WorkBuddy 写脚本(钩子+知识点+金句):
帮我写一条 60 秒的口播短视频脚本,主题:为什么长跑并不适合所有人,要求:开头有悬念、中间有知识点、结尾有金句,语气轻松但专业,字数约 200 字
3-8分钟:生成配图
根据脚本内容,生成4-6张统一风格的配图:
根据上面的脚本,帮我生成 5 张配图,统一使用清新扁平插画风格,灰蓝色调,每张图对应脚本的一个段落
每张图消耗约5-10积分,5张图总计约50积分。图片十几秒就能出一张,快速迭代到满意。
8-18分钟:关键图生视频
选择最关键的1-2张图,让它们动起来:
用第 3 张配图(闹钟和床的画面),生成一个短视频:闹钟在床头柜上震动,被子微微起伏,清晨微光透过窗帘,慢动作,竖屏
视频生成约2-5分钟,消耗约50-100积分/条。建议只对最关键的画面生成视频,其他用静态图配字幕即可。
18-28分钟:批量合成
让 WorkBuddy 用 FFmpeg 批量合成:
帮我把这些图片和视频合成一个 60 秒竖屏视频,每张图配对应音频,加底部字幕,保存到桌面
WorkBuddy 会生成 FFmpeg 命令,直接批量合成,不需要你手动剪辑。
28-30分钟:导出成片
60秒视频,5个场景,有人物、有知识点、有转折、有金句。全程耗时约30分钟(含人工调整)。如果不追求完美,20分钟就能出一条。
七、避坑指南(高频QA)
避坑指南
画面不对 → Prompt太虚,加细节或先出图验证
手畸形 → 否定描述加上,源图手要正常
生成超时 → 等会重试,最多1次,再简化Prompt
商用风险 → 自媒体一般OK,广告建议人工审核
人物不一致 → 固定角色描述关键词,每次生图都加上
工具是杠杆,用力靠人。WorkBuddy 没有"替代你做视频",而是把门槛刨平了——你不再需要全会拍、剪、配、写,只要会描述、懂工作流、能判断。差别永远在:谁的Prompt更准、谁更省、谁把AI和人工结合得更巧。
如果你也想30分钟做出一条自媒体短视频:
WorkBuddy 是腾讯出品的职场 AI 智能体,视频生成只是它几十个技能里的一个。扫码注册,用 3qevy0z9g3umcxzx 这个邀请码,我们一起把4.5小时的制作流程压缩到30分钟:

免费注册 WorkBuddy →
作者声明:本作品含 AI 生成内容。信息来源:今日头条@尘染风沙(https://www.toutiao.com/article/7685215309858488832/)。